AIBase
首頁
AI 資訊
AI 產品庫
GEO 平台
MCP 服务
模型算力廣場
VIP會員
TW

AI資訊

查看更多

Meta 首個實時音頻感知模型來了:20 多人同時說話也能分軌轉寫,每千分鍾 3 美元

Meta推出首個實時音頻感知模型Muse Voice Transcribe,可通過Model API調用,定價每1000分鐘3美元(約每小時0.18美元)。該模型整合流式語音識別、說話人分離與端點檢測,支持邊說邊轉寫,無需等待整段音頻,並可自動區分20餘名說話者分軌輸出。

17.8k 7 小時前
Meta 首個實時音頻感知模型來了:20 多人同時說話也能分軌轉寫,每千分鍾 3 美元

模型

查看更多

kimi-thinking-preview

Moonshot

kimi-thinking-preview

$200

輸入tokens/百萬

$200

輸出tokens/百萬

131

上下文長度

MCP

查看更多
NijiVoice

NijiVoice

NijiVoice-MCP是一個開發中的項目,實現了與にじボイス(Niji Voice)API的Model Context Protocol (MCP)集成,使LLM能夠通過MCP接口輕鬆調用にじボイ斯的語音合成功能,包括語音生成、聲優列表獲取和餘額查詢等。

python
10.9k
2.5分
AIBase
智啟未來,您的人工智能解決方案智庫
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商務合作網站地圖